MedScope: A Lightweight Benchmark of Open-Source Large Language Models for Medical Question Answering
O artigo apresenta o MedScope, um benchmark leve e de código aberto que avalia sistematicamente modelos de linguagem de grande porte open-source em perguntas médicas de múltipla escolha, revelando heterogeneidade significativa em desempenho e eficiência e destacando a necessidade de avaliações multidimensionais antes da implementação em cenários clínicos de alto risco.